0.25秒识破未见攻击,这套检测方法没看过任何越狱样本 | EMNLP'26 0.25秒识破未见攻击,这套检测方法没看过任何越狱样本 | EMNLP'26 关键词: AI新闻,模型训练,Learning to Detect,人工智能 大视觉语言模型(LVLM)把语言理解扩展到了图像等多模态输入,同时,也带来了更隐蔽的攻击面。 来自主题: AI技术研报 5433 点击 2026-09-03 09:50